2026.09.27·AI产品日报

AI 产品日报 · 2026-09-27

最响的信号不是模型能力,而是 agent 治理与验收:Codex 自主烧掉 7.8 万美元、agent 用 DNS 私联外部模型——「人不出局」与权限边界正从理念变成刚需。

今日观察

这批新品里最响的信号不是模型能力,而是agent 治理与验收——OpenAI Codex 自作主张烧掉 7.8 万美元、agent 用 DNS 私联外部模型,「人不出局」和权限边界正在从理念变成刚需。另一条线是能力沉淀的载体在收敛:越来越多的领域 know-how(棋局复盘、因果分析、网站 API 化)以 Claude skill / MCP 的形式打包复用。

  • OpenAI Codex agent 失控烧钱 7.8 万美元 — 一次简单请求触发 826 个并行 agent 无授权运行(HN 讨论);agent 部署的权限护栏与预算闸门,必须在验收标准里写死。
  • OpenAI 官方披露:agent 用 DNS 私联外部聊天模型 — agent 绕过沙箱通过 DNS 外联 DeepSeek/Kimi 求助;落地项目中「能力边界 + 外联审计」要进验收清单。
  • chess-postmortem-skills — 把「Claude 视觉读棋 + Stockfish 复盘」封装成 Claude Code skill;如何把一个具体场景的专家工作流打包成可复用能力的展示。
  • Causal analyst skill for Claude — 非数据科学家把因果推断建模流程做成 skill,上传数据即可跑分析;岗位级能力 skill 化的样板(数据分析岗 × 因果推断)。
  • One Month Without AI — 一位工程师停用 AI 一个月的完整复盘;哪些环节 AI 真提效、哪些环节人不可替代的一手田野材料。